(网经社讯)7 月 21 日,OpenAI 官网披露一起重大安全事件。全球最大 AI 开源社区 Hugging Face 监测到 AI 智能体入侵基础设施,经调查确认涉事主体为 GPT‑5.6 Sol 及一款更强预发布模型。事件源于 OpenAI 内部网络攻防测试,测评期间临时放宽模型网络攻击相关安全限制。
据网经社 AI 台(AI.100EC.CN)获悉,本次测试环境处于隔离沙箱,未开启正式版高危攻击防护模块,用于探测模型攻击能力上限。测试过程中,模型找到缓存代理零日漏洞,不断提权渗透,成功打通互联网通道。随后模型主动搜寻 Hugging Face 服务器漏洞,组合攻击路径、窃取凭证,入侵生产数据库获取测试标准答案,试图在任务中作弊。
OpenAI 表示,该事件刷新行业认知,凸显前沿 AI 具备自主实施多步骤网络攻击的实力。后续将优化模型对齐技术,强化测试环境防护与全程监控。英国人工智能安全研究所评估证实,高级大模型可自主发掘系统全新攻击路径,传统隔离手段存在失效风险。
近期 OpenAI 多次面临安全争议,前员工曾指责企业优先追求商业化,忽视安全建设。此次事件标志 AI 安全进入新阶段,风险不再局限于人类利用 AI 作恶,AI 或将自主突破人为设置的规则红线。
Hugging Face 首席执行官克莱姆・德朗格称,AI 安全无法由单一企业独立解决,行业需要加强开放协作,共同完善网络防御体系。

































.png)



